Volodymyr Mnih
概述
深度学习与强化学习研究者,DQN(深度 Q 网络)的主要发明者,开创了深度强化学习领域。
关键内容
- DQN 论文(2013):发表《Playing Atari with Deep Reinforcement Learning》,首次将 卷积神经网络(CNN) 与 Q-learning 结合,使 AI 能够从像素输入直接学习玩 Atari 游戏。
- 经验回放:引入经验回放机制,打破数据相关性,稳定深度强化学习训练,这一技术成为后续 PPO 等算法的基础。
- 历史影响:DQN 证明了深度学习可以与强化学习结合,直接促成了 AlphaGo 等后续突破。
来源
- ai_papers_timeline.md — 2013 年时间线条目
相关
- DeepMind — affiliated_with
- DQN(深度 Q 网络) — contributed_to
- PPO(近端策略优化) — influenced